谷歌DeepMind负责人卡武克奥卢在AI峰会透露,新一代旗舰模型Gemini 4即将推出,目前已进入后训练初期,该阶段用于提升模型行为可靠性。谷歌跳过3.5 Pro,直接押注Gemini 4,计划远早于年底发布,正加速拿出早期成果。
谷歌与DeepMind研究人员9月16日成立DeepMind研究院,旨在推动通用人工智能(AGI)跨学科讨论。董事包括Shane Legg、James Manyika、Demis Hassabis,Legg任执行主编。研究院强调呈现谷歌、DeepMind及全球研究界的不同观点,首批发布四篇文章,聚焦AGI经济政策、模型推理透明度、人类繁荣原则及前沿AI。
英国AI初创公司Emulate启动新一轮融资,目标最高7亿美元,投后估值约37亿美元,Index Ventures等领投。公司成立于2026年8月,创始人曾任职谷歌DeepMind,参与开发Genie世界模型,可据简短提示生成逼真视频与交互式3D环境,发布时引发游戏行业震动。
AI行业就AGI是否到来展开论战:黄仁勋称OpenAI推出Astra标志AGI已至;DeepMind首席AGI科学家Shane Legg公开反驳,认为当前谈AGI时代言之过早,并指出按OpenAI章程中的AGI定义衡量尚未实现。
Veo 4 是 Google DeepMind 的 AI 视频生成与图像编辑平台。
Google DeepMind旗舰多模态AI,1M上下文,具备博士级推理与高级编码能力
Nano Banana 2 是由 Google DeepMind 开发的专业 AI 图像编辑器。
Google DeepMind推出的最先进的AI天气预报技术。
Google
-
输入tokens/百万
输出tokens/百万
上下文长度
$0.14
$0.28
131
$1
$17.5
$70
2.1k
brittlewis12
Gemma 3 4B IT GGUF 是 Google DeepMind 推出的轻量级开源语言模型,基于与 Gemini 模型相同的研究和技术构建。该模型具有 128K 的大上下文窗口,支持超过 140 种语言,采用 GGUF 格式便于在各种设备上部署运行。
Gemma 3 1B IT GGUF 是 Google DeepMind 开发的轻量级开源语言模型的 GGUF 格式版本。该模型基于 Gemma 3 1B IT(指令微调)模型转换而来,具有 128K 的大上下文窗口,支持超过 140 种语言,适合在资源有限的环境中部署。
Crystalcareai
GemMoE 是基于 Deepmind 的 Gemma 架构的专家混合(MoE)模型,融合了 8 个单独微调的 Gemma 模型,每个令牌配备 2 个专家,功能强大且易于训练和推理。
HuggingFaceM4
IDEFICS是Deepmind开发的闭源视觉语言模型Flamingo的开源复现版本,支持多模态输入(图像+文本)并生成文本输出。
IDEFICS 是 Deepmind 开发的闭源视觉语言模型 Flamingo 的开源复现版本,是一个多模态模型,可以接受任意序列的图像和文本输入,并生成文本输出。
IDEFICS是一个开源的多模态模型,能够处理图像和文本输入并生成文本输出,是Deepmind Flamingo模型的开源复现版本。
IDEFICS-9B是一个90亿参数的多模态模型,能够处理图像和文本输入并生成文本输出,是Deepmind Flamingo模型的开源复现版本。
deepmind
基于BERT的掩码语言建模任务预训练,支持处理UTF-8字节输入的多模态Transformer模型
基于ImageNet预训练的通用视觉感知器模型,采用卷积预处理和Transformer架构,支持图像分类任务
基于ImageNet预训练的通用视觉感知器模型,采用学习型位置嵌入处理图像输入
oandreae
该模型是基于deepmind/language-perceiver在financial_phrasebank数据集上微调的金融文本情感分类模型。
Perceiver IO是一种通用Transformer架构,可处理多种模态数据,本模型专为图像分类任务设计,在ImageNet数据集上预训练。